중국 AI 대모델 경쟁에 다크호스 등장: StartLux
천단위(陳天橋)가 설립한 StartLux가 첫 모델인 27B 파라미터의 로컬 모델로 CAICT MCP 벤치마크에서 종합 2위를 차지했다. 1.6조 파라미터의 DeepSeek-V4-Pro와 격차는 불과 1.3%포인트에 불과하며, 클라우드 없이 소비자용 PC에서 직접 실행 가능한 점이 핵심이다. 파라미터 경쟁이 아닌 '작고 아름다운' 로컬 모델 상용화 전략이 주목받는 사례다.
천단위(陳天橋)가 설립한 StartLux가 첫 모델인 27B 파라미터의 로컬 모델로 CAICT MCP 벤치마크에서 종합 2위를 차지했다. 1.6조 파라미터의 DeepSeek-V4-Pro와 격차는 불과 1.3%포인트에 불과하며, 클라우드 없이 소비자용 PC에서 직접 실행 가능한 점이 핵심이다. 파라미터 경쟁이 아닌 '작고 아름다운' 로컬 모델 상용화 전략이 주목받는 사례다.
퍼플렉시티가 로컬 모델, 하네스(harness), 샌드박스, 커넥터를 하나로 묶은 '포터블 컴퓨터(Portable Computer)'를 엔비디아 DGX Spark 하드웨어에서 구동되는 통합 시스템으로 출시했습니다. 로컬에서 실행되는 단계에는 토큰당 비용이 발생하지 않으며, OS 수준의 샌드박스로 보안성을 강화한 점이 핵심입니다.
최근 공개된 오픈소스 AI 모델들을 개인 PC에서 직접 구동하는 환경이 비약적으로 발전하여, 코딩 등의 실무 작업에서 유의미한 결과를 내고 있습니다. 저자는 최신 Gemma 4 모델을 활용해 클라우드 API 모델의 75% 수준의 성능과 속도를 보여주는 에이전틱 코딩(agentic coding)을 로컬로 성공적으로 수행하고 있다고 강조합니다. 이는 고성능 AI를 로컬 환경에서 자율적으로 활용할 수 있는 새로운 이정표를 제시한다는 점에서 매우 중요합니다.
해커뉴스에서 클로드나 GPT 대신 로컬 AI 모델을 실제 일상 코딩에 적용한 사례를 묻는 질문이 올라왔습니다. 질문자는 단순한 테스트용이 아닌 메인 개발 도구로 완전히 전환한 사용자들의 환경 세팅과 토큰 생성 속도(tok/s) 등 성능 정보를 공유해달라고 요청했습니다. 개발자들의 실무 적용 사례를 통해 상용 API를 대체할 수 있는 오픈소스 모델의 현재 성능과 한계를 파악하는 데 도움이 되는 중요한 스레드입니다.
오픈소스 Mac 메뉴바 앱 AgentHandover가 로컬 Gemma 4(Ollama)로 화면을 관찰해 반복 워크플로를 구조화된 Skill 파일로 자동 생성합니다. MCP를 통해 Claude Code, Cursor 등 어떤 에이전트든 즉시 연동 가능하며, 전 과정이 온디바이스에서 암호화되어 처리되어 프라이버시가 강력합니다.